36氪
08-05 07:01
Kimi K3与DeepSeek V4之间,隔着原生多模态的时间差
📌 一句话:Kimi K3以原生多模态架构领先,DeepSeek V4仍采用传统拼接路线,两者差距实质是技术路线选择的结果。
💡 3个要点
架构决定上限:原生多模态从预训练阶段就融合图像与文本,拼接方案只能在表层做对齐,天花板更低
体验差距明显:Kimi K3能原生理解图表、PPT、视频内容,DeepSeek V4在复杂视觉任务上仍需"翻译"转文字处理
路线无对错:DeepSeek选择更务实的工程路线,牺牲天花板换取了更快的迭代速度和更低成本
📖 背景
国产大模型竞争进入深水区,Kimi(月之暗面)与DeepSeek(深度求索)分别代表了两种不同的多模态技术路线,近期产品发布节点接近,引发行业对比。
💭 点评
原生多模态不是营销概念,而是决定AI能否真正"看懂世界"的核心能力。DeepSeek的工程务实值得尊重,但技术账终归要还——当应用场景从对话走向复杂任务时,架构缺陷会被无限放大。这场时间差,短则半年,长则一代产品。追赶者得加速了。 ---
📡 来源:36氪
📖 原文链接
点击阅读原文 →